اقرأ المشاعر الكامنة خلف فيديو من دقيقتين.
سجّل نفسك وأنت تجيب عن خمسة أسئلة قصيرة. يُحلَّل الصوت وحركة الوجه معًا، ثم تُترجم النتيجة إلى أربعة مؤشرات وجدانية — بخصوصية تامة وخلال ثوانٍ.
- الوسائط
- 2 الوسائط
- فئات المشاعر
- 8 فئات المشاعر
- عينات التدريب
- 2,452 عينات التدريب
كيف يعمل
ثلاث خطوات وتسجيل واحد قصير
لا شيء لتثبيته ولا استمارات لتعبئتها. سجّل، وانتظر، ثم اقرأ التحليل التفصيلي.
التسجيل
أجب عن خمسة أسئلة موجّهة أمام الكاميرا. لا يغادر المقطع حسابك.
التحليل
تُقيّم ثلاث شبكات مدرَّبة الكلام وحركة الوجه والدمج بينهما.
النتيجة
اطّلع على توزيع المشاعر ودرجات المؤشرات وكيف صوّتت كل وسيلة.
داخل النموذج
شبكتان ونتيجة مدموجة واحدة
تتنبأ شبكة الكلام وشبكة الفيديو ثلاثية الأبعاد كلٌّ منهما بالمشاعر على حدة، ثم تُدمج سماتهما واحتمالاتهما في متجه واحد بـ 568 بُعدًا تحوّله شبكة الدمج إلى التوزيع النهائي.
الصوت
شبكة التفافية + BiLSTM + RNN فوق أطياف log-Mel
الفيديو
ResNet3D r3d_18 فوق مقاطع من 16 إطارًا
الدمج
شبكة MLP فوق متجه الدمج بـ 568 بُعدًا
من التسجيل إلى المؤشر
-
1
استخراج الصوت
ffmpeg → 16 kHz mono WAV
-
2
تقييم الكلام
128-band log-Mel → CNN + BiLSTM + RNN
-
3
تقييم حركة الوجه
16 frames @ 112 px → ResNet3D r3d_18
-
4
دمج الإشارتين
568-dim vector → Fusion MLP
-
5
الترجمة إلى مؤشرات
Softmax → rule-based indicator scores
نفّذ فحصك الأول
تسجيل من دقيقتين هو كل ما يحتاجه النموذج.
ابدأ الآنهذه النتيجة ليست تشخيصًا طبيًا. يرجى استشارة مختص.